Free
多語

Vibe 3.0.23 for macOS x64

Vibe 是一款完全離線、保護隱私的語音轉錄桌機應用程式 — 搭載 OpenAI Whisper,支援近百種語言、多種輸出格式與 GPU 加速。
授權性質:開源
使用限制:請參考軟體公司網站
介面語言:多國語言
作業系統:macOS
點閱次數:66
下載次數:11
檔案大小:39.81 MB
更新時間:2026/7/17 下午1:12:38
官方網站: Vibe
軟體重點及亮點
● 完全離線處理音訊,確保機密資料不離本機,有效保障使用者隱私安全。 ● 支援 NVIDIA 等硬體加速,大幅提升轉錄速度,讓繁重的語音轉換工作更順暢。 ● 內建說話者辨識功能,自動區分不同發言者,讓複雜對話的逐字稿整理更清晰。 ● 可直接從影音平台擷取音訊並轉錄,無需額外下載,讓內容創作與研究更高效。 ● 提供多種輸出格式與開源免費授權,無任何隱藏費用,滿足各種專業應用需求。
軟體簡介
你有沒有遇過這種情況——手邊有一堆會議錄音、採訪錄音或上課錄影,想要把它們轉成文字,但又不想把檔案上傳到雲端、不想付每分鐘幾塊錢的轉錄費、更不想讓第三方公司知道你說了什麼?Vibe 就是為了解決這個問題而生的。它是一款完全在本地端執行的語音轉錄工具,背後用的是 OpenAI 開源的 Whisper 模型,但你的音訊檔案不需要離開你的電腦,一切都在你自己的機器上處理完成。無論你用的是 Mac、Windows 還是 Linux,Vibe 都有相對應的版本,而且支援 NVIDIA、AMD、Intel 等各家 GPU 加速,讓轉錄速度飛快。它的介面設計得相當清爽直覺,拉個檔案進去、選好語言、點一下按鈕,轉錄稿就出來了。 支援匯出 SRT、VTT、TXT、PDF、JSON、DOCX 等格式,甚至能直接從 YouTube 連結抓音訊來轉,對內容創作者、記者、研究生、聽障人士來說都超級實用。而且它完全開源、MIT 授權、免費使用——沒有試用期、沒有浮水印、沒有用量限制。
其他版本軟體 / 作業系統

詳細說明介紹

功能特性

  • 完全離線運作:採用 OpenAI Whisper 模型,所有語音辨識都在本機執行,不需網路連線,音訊檔案不會離開你的電腦,隱私零妥協
  • 支援近百種語言:可辨識並轉錄幾乎所有主流語言,包含繁體中文、簡體中文、英文、日文、韓文、法文、德文、西班牙文等,並支援跨語言翻譯成英文
  • 多種輸出格式:支援 SRT、VTT、TXT、HTML、PDF、JSON、DOCX 等格式,滿足字幕製作、文稿整理、資料分析等不同需求
  • GPU 硬體加速:針對 macOS(CoreML)、Windows 與 Linux(Vulkan)進行 GPU 優化,支援 NVIDIA、AMD、Intel 顯示卡,大幅縮短轉錄時間
  • 批量大量處理:可一次拖入多個音訊/影片檔案進行批量轉錄,不需逐一操作
  • YouTube 與影音網站支援:直接貼上 YouTube、Vimeo、Facebook、Twitter 等平台的網址,即可下載音訊進行轉錄
  • 說話者辨識:內建 Speaker Diarization 功能,自動區分不同說話者,在轉錄稿中標示誰說了什麼
  • 即時預覽與編輯:轉錄過程中可即時預覽逐字稿,並在完成後直接編輯修正
  • AI 摘要與分析:可整合 Claude API 或本機 Ollama,對轉錄內容進行摘要、翻譯或其他 AI 分析
  • 麥克風即時錄音轉錄:直接從系統音訊或麥克風錄音並即時轉錄
  • HTTP API 與 CLI 支援:提供 Swagger 檔案化的 HTTP API 伺服器模式,以及命令列介面,適合開發者整合到自己的工作流程中
  • 自動更新與跨平台:內建自動更新機制,支援 macOS、Windows、Linux 三大桌面平台,並提供 .dmg、.deb、.rpm、.AppImage 等多種安裝格式

使用場景

  • 記者與採訪工作者:錄下採訪內容後,直接拖進 Vibe 轉成文字稿,省去邊聽邊打的痛苦,還可匯出 SRT 給影片上字幕
  • 研究生與學術研究者:將課堂錄音、演講錄影或焦點團體訪談轉錄為逐字稿,方便後續編碼分析與引用
  • 內容創作者與 YouTuber:從自己的影片或參考影片中提取逐字稿,快速產出字幕檔(SRT/VTT),提升影片可及性與 SEO
  • 聽障人士與無障礙需求:將沒有字幕的影片或會議錄音轉成文字,確保資訊平等取得
  • Podcast 製作人:將每集節目轉錄為文字稿,放在官網上作為 show notes,改善搜尋引擎排名與聽眾體驗
  • 會議記錄與商業應用:內部會議、客戶訪談結束後快速產出逐字會議記錄,且因完全離線處理,機密資訊不會外洩
  • 語言學習者:將外語音訊轉錄為文字,搭配翻譯功能輔助理解,或製作雙語對照字幕

系統基本需求

  • 作業系統:macOS(Intel 與 Apple Silicon)、Windows(10/11,x86_64 與 ARM64)、Linux(x86_64 與 ARM64,支援 .deb、.rpm、.AppImage)
  • 記憶體:基本需求 4GB 以上;建議 8GB 以上以順暢執行大型 Whisper 模型
  • 儲存空間:軟體本體約 40MB;Whisper 模型檔案約 150MB(tiny)至 3GB(large-v3),依選擇模型而定
  • GPU:非必要但建議具備。支援 NVIDIA(CUDA/Vulkan)、AMD(Vulkan)、Intel(Vulkan)與 Apple(CoreML)GPU 加速
  • CPU:支援 AVX2 指令集可獲得最佳效能;ARM 架構(Apple Silicon、樹莓派)亦可執行
  • 網路連線:初次使用需下載 Whisper 模型;後續離線轉錄不需網路。若使用 YouTube 轉錄或 Claude/Ollama 功能則需網路

免費資訊

  • 完全免費且開源,採用 MIT 授權條款。無付費版本、無訂閱制、無浮水印、無用量限制。原始碼完整公開於 GitHub,社群活躍,持續更新維護中。若喜歡此專案,可透過 GitHub Star 或贊助方式支援開發者。

多國語言介面

  • 應用程式本身的使用者介面已內建多國語言支援,社群貢獻了包括英文、繁體中文、簡體中文、日文、韓文、法文、德文、西班牙文、葡萄牙文、俄文等多種語言的翻譯檔。可透過修改語言設定檔輕鬆切換。轉錄功能方面,Whisper 模型本身支援近百種語言的語音辨識。

總結

  • Vibe 是那種「用了就回不去」的轉錄工具。市面上不是沒有其他選擇——Google 有語音轉文字 API、Otter.ai、Sonix 之類的服務也很成熟——但那些全是雲端服務,你得把音訊檔上傳給別人,還得按時付費。Vibe 把所有東西都搬到了你的電腦上,速度不輸雲端服務,隱私卻完全在你的掌控之中。它的使用體驗也做得相當到位:介面設計簡潔美觀、操作邏輯直覺流暢、支援的輸出格式應有盡有。雖然大型 Whisper 模型在沒有 GPU 的機器上會跑得比較慢,但對於重視隱私、需要大量轉錄、或是經常有機敏內容要處理的使用者來說,Vibe 幾乎是無可挑剔的解決方案。MIT 開源授權、跨平台支援、活躍的社群開發——只能用一句話總結:佛心軟體,不裝嗎?

如果您覺得此軟體符合您的需求,請點擊下方按鈕前往下載頁面。

立即進入下載頁面

軟體截圖參考

該公司的其他軟體

資料讀取中...